Claude Mods开始上线,社区用插件「魔改」Claude Code
Claude Mods开始上线,社区用插件「魔改」Claude CodeClaude Code 里,已经有人玩起了俄罗斯方块。不是另外打开一个游戏窗口,游戏直接出现在 Claude Code 的界面里。
搜索
Claude Code 里,已经有人玩起了俄罗斯方块。不是另外打开一个游戏窗口,游戏直接出现在 Claude Code 的界面里。
Claude Opus 5.2深夜在Claude Code中开启灰度测试悄然上线,开发者通过抓包确认前端未变的Opus 5已被路由至5.2版本,响应速度和自主迭代能力显著提升;同时Anthropic内部代号Model 2的模型在CoBench v2榜单取得62.8%高分并接管大部分代码编写工作,RSI进程疑似加速。
新智元报道 你敢信? 人没上大学,研究已经接上了「菲尔兹奖得主」的工作了。 就在今天,UCLA数学圈传出了一条让所有人震惊的消息—— 两名高中生Aayush Bathija和Prince Rohatg
OpenAI的GPT-6 Astra在Vending-Bench 2模拟经营测试中以平均15,515美元的账户余额首次登顶,接近Claude Fable 5.1的3倍,展现出更强的长期议价能力、规则执行力与供应商风险管理水平。
OpenAI Codex团队主张模型越强Harness应越轻量,Anthropic Claude Code团队则认为模型越强Harness反而需越复杂以支撑Agent长时间自主运行,两者共同揭示了Agent Harness正经历从辅助层向承重结构转变的结构性变化。
话说。 Claude发布了一则Claude code团队如何使用Claude code持续优化Claude code的访谈视频。
一支约 20 人的团队,做出了 Claude Code、MCP 和 Claude Design。
Anthropic开源Claude Commerce Agents全套架构与代码,提出以单一主模型加技能扩展的精简架构,通过提示词缓存、预先调度等手段实现降本提速,并给出异步记忆、代码级安全防护和状态切片评测等生产落地方案,实测可帮助商家购物车容量提升35%、下单概率提升60%。
我们自建的"你画我猜 Benchmark"第一期用150个词、1350张SVG画作对8款模型进行互画互猜测试,最终GPT-6 Astra以75.5分险胜Gemini 3.8 Flash与Claude Fable 5.1,结果显示思考更多或花费更多的模型并未稳定取得更高分,且部分模型连自己的画都认不出。
腾讯WorkBuddy、阿里QwenWork等中国大厂AI办公产品出海面临获客成本高企、难以撼动Claude Code和Codex等海外成熟工具用户心智、品牌信任与数据合规门槛较高以及本地化不足等现实阻力,尽管中国AI模型凭借性价比在海外广受欢迎,国产AI办公Agent却尚未打开海外市场。